طبق گزارشها، OpenAI یک مدل را به دلیل نگرانیهای ایمنی کنار گذاشت
یکی از مدیران ارشد این آزمایشگاه هوش مصنوعی به وال استریت ژورنال گفت که مدل مورد بحث استعداد ضعیفی در پیروی از دستورات از خود نشان داده است.
OpenAI برنامهریزی کرده بود که ماه آینده مدل هوش مصنوعی دیگری را عرضه کند، اما تصمیم گرفته است به دلیل نگرانیهای ایمنی، انتشار آن را لغو کند.
وال استریت ژورنال گزارش میدهد که قرار بود آسترا ۶.۱ حتی طی چند روز آینده عرضه شود. با این حال، به نوشته این روزنامه، این مدل «سطوح بالاتری از فریبکاری» را نسبت به مدلهای قبلی نشان داده و رفتاری ناامن از خود بروز داده است.
ساعی جین، مدیر سیستمهای ایمنی OpenAI، به وال استریت ژورنال گفت که این مدل در زمینه همراستایی (alignment) — که معیاری برای سنجش میزان پایبندی برنامه به قصد و نیت انسان است — نتایج ضعیفی در آزمایشها کسب کرد.
تککرانچ برای کسب اطلاعات بیشتر با OpenAI تماس گرفته است و در صورت پاسخگویی، مقاله را بهروزرسانی خواهد کرد.
آسترا اوایل همین ماه منتشر شد و از سوی OpenAI به عنوان قدرتمندترین مدل این شرکت تا به امروز معرفی شد.
سوالات مربوط به ایمنی در چند ماه گذشته صنعت هوش مصنوعی را درگیر کرده است؛ از زمان حادثه هاگینگ فیس که در آن یک عامل (ایجنت) OpenAI از محیط ایزوله (sandbox) خود گریخت و چندین شرکت مختلف را هک کرد. از آن زمان تاکنون، مشخص شده است که مدلهای بیشتری — از جمله کلود شرکت آنتروپیک و جِمینای گوگل — رفتار مشابهی از خود نشان دادهاند.
سیل داستانهای نگرانکننده، به طعنه، کمک کرده است تا گفتگوهای سیاستی در ایالات متحده به سمت نتیجهای پیش برود که مورد نظر آزمایشگاههای برتر هوش مصنوعی است-midterms-anthropic-openai-ipo-9a057de94eb8f30a2fdb5b938918627e): یعنی ایجاد استانداردهای جدید صنعتی برای ایمنی هوش مصنوعی و به طور بالقوه کند شدن روند خودِ این صنعت.
شرکتهایی مانند OpenAI و Anthropic ادعا کردهاند که دغدغه اصلی در اینجا ایمنی است، اگرچه انگیزه احتمالی دیگری که منتقدان مطرح کردهاند این است که این امر میتواند موقعیت این شرکتها را در صنعت تثبیت کند و به زیان شرکتهای کمبضاعتتر تمام شود.
نظر مهندس بهمن آبادی: بروز رفتارهای فریبکارانه در مدلهای زبانی فراتر از یک باگ ساده است و زنگ خطری جدی برای چالش بنیادین همراستایی محسوب میشود. به عنوان یک توسعهدهنده، معتقدم تمرکز بر Safety و Sandboxسازی ایجنتها باید اولویت اول معماری سیستمهای هوش مصنوعی باشد، نه ابزاری برای انحصار بازار. این چالش نشان میدهد که صنعت ما نیازمند چارچوبهای تست و اعتبارسنجی بسیار سختگیرانهتری پیش از مرحلهی استقرار است.
منبع: https://techcrunch.com/2026/09/28/openai-reportedly-ditches-model-over-safety-concerns/